Micron Document
<!DOCTYPE html>
<html class="client-nojs vector-feature-language-in-header-enabled vector-feature-language-in-main-page-header-disabled vector-feature-page-tools-pinned-disabled vector-feature-toc-pinned-clientpref-0 vector-toc-not-available vector-feature-main-menu-pinned-disabled vector-feature-limited-width-clientpref-1 vector-feature-limited-width-content-enabled vector-feature-custom-font-size-clientpref-1 vector-feature-appearance-pinned-clientpref-0 skin-theme-clientpref-day vector-sticky-header-enabled" lang="de" dir="ltr"><head>
<meta charset="UTF-8">
<title>Extended UNIX Coding</title>
<meta name="viewport" content="width=device-width, initial-scale=1.0">
<link rel="icon" type="image/png" href="./_res_/favicon.png">
<link rel="canonical" href="https://de.wikipedia.org/wiki/Extended_UNIX_Coding"> <link href="./_mw_/ext.wikimediamessages.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.icons.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.search.codex.styles.css" rel="stylesheet" type="text/css">
<link href="./_mw_/skins.vector.styles.css" rel="stylesheet" type="text/css">
<meta name="ResourceLoaderDynamicStyles" content="">
<link href="./_mw_/ext.gadget.citeRef.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.defaultPlainlinks.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiCommonHide.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiCommonLayout.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiCommonStyle.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiDarkmode.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.dewikiResponsive.css" rel="stylesheet" type="text/css">
<link href="./_mw_/ext.gadget.specialSearch.css" rel="stylesheet" type="text/css">
<link rel="stylesheet" type="text/css" href="./_mw_/site.styles.css">
<link rel="stylesheet" type="text/css" href="./_mw_/noscript.css">
<link rel="stylesheet" type="text/css" href="./_res_/footer.css">
<link rel="stylesheet" type="text/css" href="./_res_/vector-2022.css">
</head>
<body class="skin--responsive skin-vector skin-vector-search-vue mediawiki ltr sitedir-ltr mw-hide-empty-elt ns-0 ns-subject page-Extended_UNIX_Coding rootpage-Extended_UNIX_Coding skin-vector-2022 action-view">
<div class="mw-page-container">
<div class="mw-page-container-inner">
<div class="mw-content-container">
<main id="content" class="mw-body">
<header class="mw-body-header vector-page-titlebar">
<h1 id="firstHeading" class="firstHeading mw-first-heading"><span class="mw-page-title-main">Extended UNIX Coding</span></h1>
</header>
<a id="top"></a>
<div id="bodyContent" class="vector-body ve-init-mw-desktopArticleTarget-targetContainer" aria-labelledby="firstHeading" data-mw-ve-target-container="">
<div id="contentSub">
<div id="mw-content-subtitle"></div>
</div>
<div id="mw-content-text" class="mw-body-content mw-content-ltr" lang="de" dir="ltr"><div class="mw-content-ltr mw-parser-output" lang="de" dir="ltr"><p><b>Extended <a href="UNIX" class="mw-redirect" title="UNIX">UNIX</a> Coding</b> (<a href="Abk%C3%BCrzung" title="Abkürzung">Abkürzung</a> <i>EUC</i>) ist eine 8-<a href="Bit" title="Bit">Bit</a>-<a href="Zeichencodierung" class="mw-redirect" title="Zeichencodierung">Zeichencodierung</a>, die vor allem für <a href="Chinesische_Sprache" class="mw-redirect" title="Chinesische Sprache">Chinesisch</a>, <a href="Japanische_Schrift" title="Japanische Schrift">Japanisch</a> und <a href="Koreanische_Schrift" class="mw-redirect" title="Koreanische Schrift">Koreanisch</a> gebraucht wird. EUC ist eine Sammelbezeichnung für verschiedene <a href="Kodierung" class="mw-redirect" title="Kodierung">Kodierungen</a>, die je nach Land bis zu vier unterschiedliche <a href="Zeichensatz" title="Zeichensatz">Zeichensätze</a> kodieren können. Ursprünglich entwickelt von der <a href="Open_Software_Foundation" title="Open Software Foundation">Open Software Foundation</a> (OSF), Unix International (UI) und den Unix System Laboratories Pacific (USLP) als Standardkodierung für UNIX-Systeme, findet diese Kodierung heute immer weniger Verwendung, da sie oft von weiter verbreiteten lokalen Kodierungen (<a href="Shift-JIS" class="mw-redirect" title="Shift-JIS">Shift-JIS</a>, <a href="Big5" title="Big5">Big5</a> etc.) und/oder <a href="Unicode" title="Unicode">Unicode</a> (<a href="UTF-8" title="UTF-8">UTF-8</a>) abgelöst wurde.
</p>

<div class="mw-heading mw-heading2"><h2 id="Gemeinsamkeiten">Gemeinsamkeiten</h2></div>
<p>Alle EUC Kodierungen haben einige Gemeinsamkeiten:
</p>
<ul><li>Sie unterstützen bis zu vier verschiedene <a href="Zeichensatz" title="Zeichensatz">Zeichensätze</a>, in EUC-Terminologie <b>Code Sets</b> genannt. Code Set&nbsp;0 ist immer (7-Bit)-<a href="American_Standard_Code_for_Information_Interchange" title="American Standard Code for Information Interchange">ASCII</a>, Code Sets 1–3 sind je nach Unterart verschieden.</li>
<li>Code Set 0 wird immer durch ein Byte direkt kodiert.</li>
<li>Es gibt zwei Spezialzeichen (<a href="Escape-Sequenz" title="Escape-Sequenz">Escape-Zeichen</a>), die zum Umschalten auf Code Set&nbsp;2 bzw. Code Set&nbsp;3 verwendet werden: SS2&nbsp;(0x8e) und SS3&nbsp;(0x8f).</li>
<li>Der Nicht-ASCII Bereich von 0xa0–0xff wird für Multi-Byte-Zeichen verwendet.</li></ul>
<p>Für die Code Sets 1 bis 3 gibt es mehrere Möglichkeiten der Kodierung (je nach Untervariante von EUC unterschiedlich). Folgende Kodierungen sind möglich:
</p>
<table class="wikitable">

<tbody><tr class="hintergrundfarbe6">
<th>Code Set
</th>
<th>Variante 1
</th>
<th>Variante 2
</th>
<th>Variante 3
</th></tr>
<tr>
<td>Code Set 0
</td>
<td>1 Byte: 0x21–0x7e
</td>
<td>
</td>
<td>
</td></tr>
<tr>
<td>Code Set 1
</td>
<td>1 Byte: 0xa0–0xff
</td>
<td>2 Bytes: 0xa0–0xff, 0xa0–0xff
</td>
<td>3 Bytes: 0xa0–0xff, 0xa0–0xff, 0xa0–0xff
</td></tr>
<tr>
<td>Code Set 2
</td>
<td>2 Bytes: 0x8e, 0xa0–0xff
</td>
<td>3 Bytes: 0x8e, 0xa0–0xff, 0xa0–0xff
</td>
<td>4 Bytes: 0x8e, 0xa0–0xff, 0xa0–0xff, 0xa0–0xff
</td></tr>
<tr>
<td>Code Set 3
</td>
<td>2 Bytes: 0x8f, 0xa0–0xff
</td>
<td>3 Bytes: 0x8f, 0xa0–0xff, 0xa0–0xff
</td>
<td>4 Bytes: 0x8f, 0xa0–0xff, 0xa0–0xff, 0xa0–0xff
</td></tr></tbody></table>
<div class="mw-heading mw-heading2"><h2 id="EUC-JP">EUC-JP</h2></div>
<p><b>EUC-JP</b> stellt die in Japan verwendete Variante dar.
</p><p>Code Set 0 ist <a href="American_Standard_Code_for_Information_Interchange" title="American Standard Code for Information Interchange">ASCII</a> (genaugenommen <a href="JIS-Roman" title="JIS-Roman">JIS-Roman</a>) und wird durch ein Byte aus dem Bereich 0x21 bis 0x7e direkt kodiert.
</p><p>Code Set 1 ist <a href="JIS_X_0208" title="JIS X 0208">JIS X 0208:1997</a> und wird durch zwei Zeichen kodiert (Variante 2 in der obigen Tabelle)
</p><p>Code Set 2 sind halbbreite <a href="Katakana" title="Katakana">Katakana</a>, die auch durch zwei Bytes kodiert werden (Variante&nbsp;1 in der Tabelle). Das zweite Byte ist hierbei allerdings nur aus dem Bereich 0xa1 bis 0xdf, da es nur 56 Katakana (und eine Handvoll Sonderzeichen) gibt und diese dann der 1-Byte Kodierung aus <a href="JIS_X_0201" title="JIS X 0201">JIS X 0201:1997</a> entsprechen (nur eben mit dem <a href="Escape-Sequenz" title="Escape-Sequenz">Escape-Zeichen</a> 0x8e als <a href="Pr%C3%A4fix" title="Präfix">Präfix</a>).
</p><p>In Code Set 3 wird <a href="JIS_X_0212" title="JIS X 0212">JIS X 0212:1990</a> in der drei Byte Variante kodiert.
</p>
<div class="mw-heading mw-heading2"><h2 id="EUC-KR">EUC-KR</h2></div>
<p><b>EUC-KR</b> ist die in Korea verwendete Version von EUC. Sie ähnelt <a href="ISO-2022-KR" class="mw-redirect" title="ISO-2022-KR">ISO-2022-KR</a> (bzw. <a href="KS_X_1001" title="KS X 1001">KS X 1001</a>).
</p>
<div class="mw-heading mw-heading2"><h2 id="EUC-CN">EUC-CN</h2></div>
<p><b>EUC-CN</b> wird in China verwendet und entspricht <a href="GB2312" title="GB2312">GB2312</a>. Es kodiert die vereinfachten chinesischen Schriftzeichen.
</p>
<div class="mw-heading mw-heading2"><h2 id="EUC-TW">EUC-TW</h2></div>
<p>Eigentlich entwickelt für Taiwan, wird <b>EUC-TW</b> nur sehr selten verwendet. Sehr viel verbreiteter ist dort <a href="Big5" title="Big5">Big5</a>. Beide kodieren die traditionellen chinesischen Schriftzeichen.
</p></div><!--htdig_noindex--><div><div class="zim-footer">
Dieser Artikel wurde von <a class="external text" title="Zuletzt bearbeitet am 2017-12-09" href="https://de.wikipedia.org/wiki/?title=Extended_UNIX_Coding&amp;oldid=171799424">Wikipedia</a> herausgegeben. Der Text ist unter <a class="external text" href="https://creativecommons.org/licenses/by-sa/4.0/deed.de">Creative Commons Attribution-Share Alike 4.0</a> verfügbar, sofern nicht anders angegeben. Für die Mediendateien können zusätzliche Bedingungen gelten.
</div>
</div><!--/htdig_noindex--></div>
</div>
</main>
</div>
</div>
</div>
<script src="./_webp_/webpHandler.js"></script>

</body></html>